前两个月,我帮一个做智慧零售的朋友做设备选型顾问。当时他从三家供应商里挑了一款AI迷你主机,理由很充分:最新的NPU、32GB内存、价格比对手低15%。结果设备铺到门店第三天就出状况——下午客流高峰,测温门禁和人脸支付频繁超时。折腾了两周才发现,那款机器在持续推理负载下散热压不住,芯片降频后算力直接打了对折。
这次经历让我意识到,AI迷你主机的批量采购,不能只看配置单。几百台设备铺下去,任何一个短板都会被放大成系统性风险。而且很多关键问题,恰恰是参数表里看不出来的。
如果你正在规划类似的采购项目,下面这六个维度,值得在签合同前逐一验证。
现在市面上的AI迷你主机,算力标注从十几到几十TOPS不等,但这些数字几乎都是理论峰值——在理想电压、理想温度、理想散热条件下跑出来的实验室数据。
真实业务场景要复杂得多。数据从内存搬到NPU内部这个动作本身就有延迟和功耗,如果模型结构里包含大量不规则访存操作,实际吞吐可能只有标称值的六成。更隐蔽的问题是算子兼容性——有些NPU对PyTorch或ONNX的某些层支持不完整,官方demo跑得通,换成你自己的业务模型就可能报错或回退到CPU。
所以最务实的做法是:采购前拿你们最核心的模型,在候选设备上完整跑一遍推理流程,看真实的QPS和延迟。如果供应商连这个测试环境都不愿意配合,后面的合作风险会比较高。
AI推理对内存的需求容易被低估。很多人觉得模型文件多大就占多大内存,但实际上,中间激活张量、KV Cache、多路并发的上下文,这些都会显著推高内存占用。
我们曾测试过一台16GB的AI迷你主机跑7B量化模型,单路推理勉强能跑,并发数稍微上来就开始频繁GC,延迟抖动明显。换到32GB版本后稳定很多。关键是,大多数迷你主机的内存是板载的,采购时没选够,后期没法升级。预算允许的话,往高配一档会更从容。
迷你主机体积小,发热密度其实很高。AI推理又是持续高负载任务,不是跑个分就结束。散热方案的好坏,直接决定了设备能不能持续跑满标称性能。
看散热不能只看有没有风扇,更要关注风道设计——进风口和出风口的位置是否合理,多台密集摆放时会不会互相影响。我们有个项目把设备放在机柜里,几十台叠放后中间那几台温度明显偏高,系统日志里频繁出现降频记录。
另外,如果设备部署在门店或办公区域,风扇噪音也是个实际问题。建议让供应商提供样机,跑负载时实际听一下噪音水平。
迷你主机为了做小体积,接口通常比较精简。但批量部署时,接口的每一项短板都会被放大。
视频输入方面,如果业务涉及人脸识别或客流动线分析,需要外接多个摄像头,那设备支持的视频输入路数和接口类型就得提前确认。有些型号只有HDMI输出,输入全靠USB摄像头,延迟和稳定性都不理想。
USB供电能力也容易出问题。外接双目摄像头、红外补光灯、加密狗这些设备后,如果主板USB口供电不足,外设会频繁掉线。采购时可以确认一下USB口的输出电流规格,优先选带独立供电设计的型号。
网络接口对于园区或工厂场景尤其重要。千兆是基础,2.5G更好,双网口在多网络隔离或链路聚合时会灵活很多。
硬件选好了,软件跑不起来,这是批量采购中最被动的局面。
不同厂商对NPU驱动和推理SDK的维护深度差异很大。有的对ONNX Runtime和TensorFlow Lite适配得很好,模型转换基本一键完成;有的则需要写大量胶水代码,甚至要手动改写算子。
建议在采购前让供应商提供同行业、同类业务的实际部署案例,看看他们是否有过类似场景的交付经验。另外,系统升级策略也值得问清楚——后续如果需要升级内核或驱动来适配新模型,厂商的响应周期和长期支持计划是怎样的。
零售和批量采购的售后逻辑完全不同。几百台设备运行,每月有一定故障率是正常的,关键在于故障后多久能恢复。
备件政策是核心。厂商是否提供备件池?故障设备是寄修还是现场更换?维修周期多长?这些都应该在合同里明确。一些有经验的供应商会提供替换机服务——你先收到备用机顶上业务,坏机再寄回去修。这种服务是否收费、响应时效如何,提前问清楚比事后沟通要主动得多。
单台设备的采购价,在批量采购中的权重其实没那么高。真正影响预算的是长期运营成本。
功耗是第一项。两台算力相近的AI迷你主机,满载功耗可能差出十几瓦。一百台设备跑一年,电费差额可能已经抵消采购价的差距了。空间利用率同样值得关注——同样算力下体积更小的设备,能帮你节省机柜租金。
最后聊聊厂商筛选。AI迷你主机赛道,有传统迷你主机厂商转型的,有AI芯片公司自己出整机的,也有ODM贴牌的。
我的经验是,优先选择有自研NPU或深度定制能力的供应商。AI推理的软件栈优化,很多时候需要芯片层面的支持才能做好。纯组装厂拿公版方案,驱动和SDK的优化深度往往不足,遇到问题时的解决能力也有限。同时可以考察一下这个厂商在你们行业是否有过批量交付记录——踩过的坑他们自己已经填平了,你跟着走会顺畅很多。